返回Model 2

Model 2

Anthropic
2026-08-18 08:03:11

SemiAnalysis称 Anthropic 已雪藏 Mythos 2,并用其数据推进 Mythos 3

SemiAnalysis 一档内部播客称,Anthropic 已完成 Mythos 2 训练,但未对外发布,当前正利用该模型生成数据和编写代码,以推进 Mythos 3。播客中,Dylan Patel 与 Jordan Nanos还提到,受安全与监管因素影响,Anthropic 和 OpenAI 均有更强模型未公开,公开版本与内部能力存在差距。报道同时援引 Anthropic 风险报告、OpenAI 内部评估及高管表态,围绕模型发布、反馈循环和安全约束展开讨论。

350
SemiAnalysis称 Anthropic 已雪藏 Mythos 2,并用其数据推进 Mythos 3
Anthropic
2026-08-16 07:57:52

Anthropic 上调失准风险评级,并披露未发布模型 Model 2

Anthropic 在 8 月 14 日发布第二份全公司风险报告,将高风险情境下因失准导致灾难性危害的风险评级从「极低」上调至「低」。公司称,此次调整并非因为模型未通过安全测试,而是近期网络安全评估事件增加了不确定性,且内部能力基准已出现「饱和」。报告还首次披露内部模型 Model 2,其能力略强于 Mythos 5,但尚未完成常规上线前评估,也暂无对外发布计划。

90
Anthropic 上调失准风险评级,并披露未发布模型 Model 2
阿里巴巴
2026-08-15 09:03:32

阿里开源 Qwen3.8-27B:14 项对比中 9 项领先 Claude

阿里巴巴于 8 月 14 日开源 Qwen3.8-27B。这是一个 270 亿参数的原生多模态模型,采用 Apache 2.0 授权,原生支持 262K 上下文,并可通过 YaRN 外推至 100 万 tokens。按阿里官方模型卡披露的 14 项对比,Qwen3.8-27B 在 9 项指标上领先 Claude Opus 4.6 Max,但落后的 5 项集中在纯推理与长链编码。4-bit 量化后约需 14 至 17GB 显存,不过这一数字不包含 KV cache 与多模态组件,目前也还没有第三方独立复现。

240
阿里开源 Qwen3.8-27B:14 项对比中 9 项领先 Claude
Anthropic
2026-08-15 01:55:08

Anthropic披露内部更强模型 Model 2,暂不计划对外发布

Anthropic在第二份《Risk Report》中首次确认,内部运行着一款强于 Mythos 5 的模型 Model 2,并称暂无对外发布计划。报告显示,Model 2 在 AECI 与 CoBench 等内部评测中高于 Mythos 5 和 Mythos Preview,同时已被大量用于编码、Agent 工作和数据生成。Anthropic还把高风险场景下的“误对齐”风险评级从“极低”上调至“低”,并承认部分基于任务的评测已出现“饱和”。

260
Anthropic披露内部更强模型 Model 2,暂不计划对外发布